AI资讯新闻榜单内容搜索-Agent

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Agent
刚刚,全球首个开源Agent会话平台发布!老板、同事和我共享一个AI

刚刚,全球首个开源Agent会话平台发布!老板、同事和我共享一个AI

刚刚,全球首个开源Agent会话平台发布!老板、同事和我共享一个AI

当 AI Agent 开始连续数小时替人工作,真正有价值的就不只是最终成果,还有藏在会话(Session)里的整个过程:它做过什么、哪里失败、为何改变方向。

来自主题: AI资讯
6912 点击    2026-09-17 10:50
Meshy: 角色驱动下SPMD范式的RL训练框架

Meshy: 角色驱动下SPMD范式的RL训练框架

Meshy: 角色驱动下SPMD范式的RL训练框架

在过去的几年里,LLM RL 系统的工作负载发生了巨大的变化。早期的 RLHF 围绕同步训练展开:模型按固定顺序进行生成、打分和训练,每个阶段之间有着明确的同步边界。如今,系统还需要处理异步生成、持续训练、多轮 Agent 以及与外部环境的交互 —— 那些在同步执行中原本隐含的状态、版本和故障边界,现在都必须显式地进行管理。

来自主题: AI技术研报
10489 点击    2026-09-17 10:11
自进化社媒Agent!浙大x北大:从多模态任务编排到反馈驱动

自进化社媒Agent!浙大x北大:从多模态任务编排到反馈驱动

自进化社媒Agent!浙大x北大:从多模态任务编排到反馈驱动

当大模型已经能够快速生成文案、图片和视频,一个更进一步的问题是:Agent 能否从执行过的任务中积累经验,并在持续交互中改进后续行为?

来自主题: AI技术研报
10087 点击    2026-09-16 14:40
复杂的Harness Evolution,甚至不如多跑几遍

复杂的Harness Evolution,甚至不如多跑几遍

复杂的Harness Evolution,甚至不如多跑几遍

一个 Agent 第一次没把任务做对。

来自主题: AI技术研报
6944 点击    2026-09-16 14:40
谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻

谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻

谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻

谷歌发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,后者支持后台异步推理与工具调用以解决语音 Agent 在任务执行中的沉默问题,两款模型已在 Gemini API 和 Google AI Studio 向开发者开放。

来自主题: AI资讯
9146 点击    2026-09-16 11:43
别让Agent瞎想乱搜还闯祸:哪些能力该内化进模型,哪些必须交给Harness,这篇讲透

别让Agent瞎想乱搜还闯祸:哪些能力该内化进模型,哪些必须交给Harness,这篇讲透

别让Agent瞎想乱搜还闯祸:哪些能力该内化进模型,哪些必须交给Harness,这篇讲透

北航、南方科技大学、复旦大学、北京理工大学、爱丁堡大学等 8 家机构的 19 位研究者联合完成 Theory of Agent 综述,讨论模型内部与外部 harness 应如何分配能力,并据此梳理 LLM Agent 的学习、对齐、演化与评测。

来自主题: AI技术研报
8904 点击    2026-09-16 10:07
Codex想让Harness消失,Claude Code却要把它做成“承重墙”

Codex想让Harness消失,Claude Code却要把它做成“承重墙”

Codex想让Harness消失,Claude Code却要把它做成“承重墙”

OpenAI Codex团队主张模型越强Harness应越轻量,Anthropic Claude Code团队则认为模型越强Harness反而需越复杂以支撑Agent长时间自主运行,两者共同揭示了Agent Harness正经历从辅助层向承重结构转变的结构性变化。

来自主题: AI资讯
9551 点击    2026-09-13 13:00
实测央企出品数字员工,它的强大远超预期!

实测央企出品数字员工,它的强大远超预期!

实测央企出品数字员工,它的强大远超预期!

实测显示,中国联通元景数字员工基于自研Agent Harness架构,具备全渠道触达与超千项技能,在深度研究、全时助理等办公场景中表现稳定可靠,并已在政务、工业、文旅等领域实现行业落地。

来自主题: AI资讯
7949 点击    2026-09-11 16:03
GPT-6 Astra,限时免费!我已爽玩

GPT-6 Astra,限时免费!我已爽玩

GPT-6 Astra,限时免费!我已爽玩

AI大模型评测平台Arena宣布用户可在直接模式中限时免费使用GPT-6 Astra(仅限medium级别),大量开发者涌入体验开发游戏,目前该模型在Agent Arena榜单中整体排名第二、前端网页开发排名第一。

来自主题: AI资讯
9841 点击    2026-09-10 15:44
V4.1 Flash全面超越,开发者为何还在喷 DeepSeek:缺的不是能力,是软件工程思维

V4.1 Flash全面超越,开发者为何还在喷 DeepSeek:缺的不是能力,是软件工程思维

V4.1 Flash全面超越,开发者为何还在喷 DeepSeek:缺的不是能力,是软件工程思维

崔添翼最近在 X 上刷屏有点多。9 月 9 日,这位今年 3 月加入 DeepSeek、负责 Agent 运行和评估基础设施的 Harness 团队成员发推称,V4.1 Flash 在性能、费用、速度和总用时等方面全面超过 V4 Pro,因此 V4.1 Flash 上线后、V4.1 Pro 上线前,所有发往 V4 Pro 的请求都会被路由到 V4.1 Flash,按 Flash 的价格计费。

来自主题: AI资讯
9924 点击    2026-09-10 15:17